ACI 设计原则
概述
ACI 设计原则是类似人机界面(HCI)的工具接口设计方法论,源自 SWE-agent 论文的四条核心原则,并在 Anthropic 工程实践中得到进一步验证和扩展,强调接口设计对 Agent 行为的决定性影响。
关键内容
原则一:动作要简单、容易理解
"Actions should be simple and easy to understand for agents."
- 很多 bash 命令太灵活、太开放、语义负担太重,对 LM 不友好
- 少量、清晰、功能边界明确的动作更好
- 背后的逻辑:语言模型对"语义上明确的工具"更容易形成稳定使用模式,而对几乎无限制的 shell 容易出现动作选择混乱
实验支撑:Shell-only baseline 对比证明,为 LM 专门设计的动作集优于原始 Linux shell。
原则二:反馈要简洁、信息密度高
"Feedback should be specific and concise."
- 人类可以忽略无关信息,但对 LM 来说所有内容都有固定 token 成本和干扰成本
- ACI 的反馈设计本质上是"压缩状态表示"——加工成足够行动、又不至于淹没上下文窗口的观察
- 这个点对今天所有 agent 仍然成立
原则三:帮助模型感知状态变化
- 好的 ACI 应该帮助 agent 理解当前状态、此前改动的后果、以及最近动作的结果
- 编辑后给出更新后的文件片段,就是"状态可见性"的例子
- 本质:把软件工程从"token continuation"变成"stateful control"
原则四:要有 Guardrails(护栏)
- Guardrails 可以减少错误传播、加速恢复
- 例如在编辑动作中加入 syntax checker
- 不是锦上添花,而是 agent 系统稳定性的核心——LM 很容易在早期引入小错误,然后整条轨迹被污染
- Guardrail 的作用是在"错误刚出现时"把它截断
Anthropic 工程实践扩展
Anthropic 在多篇文章中进一步验证和扩展了 ACI 设计理念:
-
ACI 概念起源:在 Building Effective Agents 中首次提出,将工具接口设计类比为传统的人机界面(HCI),强调接口设计对 Agent 行为的决定性影响。
-
AI 辅助工具描述改进:2025 年 9 月提出的 Writing Tools for Agents 方法,利用 AI 自我改进工具描述,实现任务完成时间降低 40%。这是 ACI 设计的自动化演进路径。
-
工具设计对 Agent 行为的影响:上下文工程研究表明,工具接口设计直接影响 Agent 的上下文使用效率和任务完成率。绝对路径案例证明微小设计差异导致显著性能差异。
-
与 MCP 的关系:MCP(Model Context Protocol)是 ACI 设计的具体实现标准,通过 Desktop Extensions 实现一键安装 MCP 服务器,降低生态系统摩擦。
-
并行工具调用与 tool_choice 控制:2025 年 11 月提出的高级工具使用模式,支持并行执行和精确控制,是 ACI 设计的高级形态。
实验验证
论文通过 消融实验 验证了这些原则: - 总结式搜索优于迭代式搜索(原则二:反馈简洁) - 100-line viewer 优于太小或全文件(原则二:信息密度) - Edit + linting 优于无 linting(原则四:Guardrails) - 最近 5 条 observation 优于 full history(原则二:简洁反馈)
来源
- raw/ChatGPT-Chat/ChatGPT-SWE-agent 论文核心观点/03-SWE-agent 论文的所有核心概念 展开详细分析 一个一个.md — SWE-agent 核心概念分析
- raw/ChatGPT-Chat/ChatGPT-SWE-agent 论文核心观点/04-SWE agent 如何保证 搜索是否高效、编辑是否稳定、反馈是否足够、上下文是否可控、恢复机制是否.md — SWE-agent 五大保障机制分析
- raw/articles/ai-engineering/anthropic-engineering/claude-engineering/00_INDEX.md — 跨文章核心主题:工具接口设计(ACI)
相关
- Agent计算机接口 — part_of(ACI 设计原则是 ACI 研究的方法论核心)
- Guardrails — extends(原则四的具体实现)
- LM Agent — uses(这些原则服务于 LM Agent 的有效行动)
- 环境反馈设计 — extends(原则二"反馈简洁高密度"的具体实现)
- 状态变化感知 — extends(原则三"状态可见性"的具体实现)
- 恢复机制 — extends(原则四"护栏机制"的恢复策略实现)
- Anthropic — part_of
- Agent 架构与设计原则 — part_of
- MCP — compares_to
- 上下文工程 — relates_to